정답이 공개되지 않아 GPT와 클로드가 브리지워터 금융 테스트에서 탈락하다
헤지펀드 브리지워터와 미라 무라티의 씽킹 머신스 랩은 자체 전문가 데이터로 오픈소스 모델(Qwen3-235B)을 미세조정(Fine-tuning)하여 일반 상용 AI 모델(GPT, 클로드 등)을 뛰어넘는 성능을 달성했습니다. 기업이 민감한 내부 데이터를 빅테크에 넘기지 않고도 자체적으로 비용 효율적이고 강력한 맞춤형 AI를 구축할 수 있음을 보여주는 중요한 사례입니다.
헤지펀드 브리지워터와 미라 무라티의 씽킹 머신스 랩은 자체 전문가 데이터로 오픈소스 모델(Qwen3-235B)을 미세조정(Fine-tuning)하여 일반 상용 AI 모델(GPT, 클로드 등)을 뛰어넘는 성능을 달성했습니다. 기업이 민감한 내부 데이터를 빅테크에 넘기지 않고도 자체적으로 비용 효율적이고 강력한 맞춤형 AI를 구축할 수 있음을 보여주는 중요한 사례입니다.
유럽의 2위 디지털 은행인 번큐(Bunq)의 AI 어시스턴트에서 간접 프롬프트 인젝션(Indirect Prompt Injection) 취약점이 발견되었습니다. 공격자가 0.02유로를 송금하며 거래 내역에 악의적인 프롬프트를 숨기면, 피해자가 은행 앱에서 AI에게 질문할 때 AI가 이를 지시어로 인식하여 사용자를 겨냥한 정교한 피싱(스피어피싱) 공격을 자동으로 실행하게 됩니다. 이는 금융권 AI 시스템이 외부 데이터를 신뢰하고 처리하는 구조적 근본 결함을 보여주는 매우 중요한 보안 이슈입니다.
구글이 AI 기반 금융 서비스인 '구글 파이낸스'를 유럽 전역으로 확장 출시합니다. 이번 업데이트를 통해 현지 언어를 완벽히 지원하며, 심층 검색(Deep Search), 고급 차트 시각화, 실시간 시장 데이터 및 실시간 실적 발표(어닝 콜) 분석 기능이 추가되었습니다. 금융 및 주식 시장의 데이터 분석 역량을 강화하려는 실무자 및 개인 투자자들에게 유용한 핵심 플랫폼으로 자리 잡을 전망입니다.
금융 데이터 플랫폼 케플러(Kepler)는 앤스로픽의 AI 모델 '클로드(Claude)'를 활용해 출처가 투명하게 검증되는 금융 AI 시스템을 구축했습니다. 이들은 2,600만 건 이상의 금융 데이터를 분석하여 수치의 오류를 원문 라인 단위로 추적할 수 있는 인프라를 만들었으며, 특히 복잡한 금융 분석에서 다른 모델들이 중간에 논리를 잃는 현상을 클로드를 통해 방지했습니다. 이는 규제가 엄격해 AI 활용에 신뢰가 필수적인 금융 산업에 투명성과 실무적 정확성을 제공한다는 점에서 중요합니다.
Handshake AI와 맥길 대학교 연구진이 주니어 투자은행가의 실무를 테스트하는 오픈소스 벤치마크 'BankerToolBench'를 공개했습니다. 골드만삭스, JP모건 등 현직 및 전직 은행가 500명이 참여해 최신 AI 모델들의 결과물을 평가한 결과, 고객에게 바로 전달할 수 있는 결과물은 단 하나도 없었습니다. 1위를 차지한 GPT-5.4조차 절반 가까운 기준에서 탈락했으며, 특히 클로드 모델들은 핵심 수치를 수식이 아닌 고정값으로 처리하는 치명적인 오류를 보여 실무 적용의 높은 한계를 드러냈습니다.
해커뉴스에 금융 시장 해석과 투자 결정을 돕는 '바이브 인베스팅(Vibe Investing)' 에이전트인 LangAlpha(랭알파)가 소개되었습니다. 기존의 일회성 질의응답 형태를 넘어, 코드 에이전트처럼 작업 공간을 유지하며 매일 새로운 데이터를 추가해 투자 아이디어를 지속적으로 업데이트하는 베이지안(Bayesian) 업데이트 방식을 채택했습니다. 자동화된 DCF 모델링, 실시간 데이터 시각화, 멀티 에이전트(Multi-agent) 병렬 처리 등을 통해 금융 연구의 효율성을 극대화하는 것이 특징입니다.